第09章 自动运营:任务、轮次与验收
把任务交给 AI 之后,它到底是怎么"排班干活"的?这一章带你看懂任务、时间片、轮次、重排、验收和人工节点——全书最核心的一章。
前面几章你已经完成了三件事:建好了公司、创建了项目、给项目配好了运行模式和预算(第 04 章),甚至已经通过智能体中心建好了几个 AI 员工(第 08 章)。现在,你站在整个平台最关键的一道门前——让 AI 真正开始"上班"。
很多新手的直觉是:给 AI 下一条大指令,等它几天后交活。真跑起来你会发现完全不是这样。AI 需要一套排班制度:谁先干、干多久、干完怎么交接、干砸了怎么办、钱不够了怎么刹车。这套制度,就是本产品里最硬核、也最值钱的一块能力——自动运营(英文叫 auto-ops)。
把项目想象成一家 24 小时开工的小工厂。厂里有几台机床(任务),有一张挂在墙上的排班表(时间片),工人每上一"班"就照表干活(轮次)。每班结束,工头会把"这班干了啥、还剩啥"写进交接本(任务接力),下一班接着干。干完一件活,不能自己说"我干好了",得交给独立质检员(验收)。遇到要老板签字的活(人工处理节点),就贴张单子等你。厂子空了就"待工省电"(空闲等待)。钱快花超了就拉闸(预算熔断)。
这一章,我们就把这张排班表从里到外看一遍。看完你就能既让 AI 高效干活,又不会让它瞎烧钱。
你将学会
- 看懂自动运营控制台上的每个按钮和数字,知道何时该点「启动」「暂停」「恢复」
- 会写一条合格的任务,并用「时间片权重」控制 AI 在一件事上花多少精力
- 理解轮次与任务接力,知道 AI 为什么能"接着上一轮继续干"
- 看懂 review 重排和空闲等待,并知道怎么把项目从"待工"状态唤醒
- 理解三权分立验收和人工处理节点,知道"什么算做完"该写在哪里
一、自动运营控制台:你的工厂总控室
自动运营控制台是这套机制的"仪表盘+总开关"。所有关于排班、预算、状态的实时信息,都汇聚在这一页。
1.1 顶部的六个按钮
打开控制台,最上方一排按钮就是你的"总开关"。它们的含义如下:
| 按钮 | 点下去会发生什么 | 什么时候用 |
|---|---|---|
| 启动 | 为这个项目拉起独立的自动运营循环,AI 开始按排班表干活 | 项目刚配好,或暂停后要重新开工 |
| 暂停 | 发出暂停信号,当前这一轮跑完才进入等待(不打断正在干活的子进程,避免丢上下文) | 临时要改方向、要开会、暂时不想让它跑 |
| 恢复 | 从下一轮继续,保留已有排班和任务接力信息 | 暂停后想接着原来的进度干 |
| 停止 | 停止循环并强停当前轮,状态置为「已停止」,服务重启也不会自动拉起 | 这个项目暂时封存,不想它再自动跑 |
| 终止项目 | 把项目置为"终止态",并生成一份结项报告 | 项目做完了、或决定彻底不做了 |
| 刷新 | 重新拉取当前页数据 | 想立刻看到最新状态 |
另外左上角还有一个 返回项目,回到项目主页。这几个按钮都会弹确认框,其中「停止」的确认文案是——
而「终止项目」会弹一个输入框,提示:请输入终止原因(将置终止态并生成结项报告)。终止是不可逆的,想清楚再点。
暂停是"先歇一会儿",循环还在,随时能「恢复」;停止是"收工",服务重启都不会自己跑起来,要重新「启动」。日常临时改东西用暂停,长期不跑用停止。
1.2 四张状态卡片
按钮下方是四张卡片,一眼看清项目"现在什么状态、花了多少钱":
运行模式
显示当前是全自动、半自动还是人工审核。旁边有 修改 按钮,点开可临时调整。
自主级别
显示 L0~L3,默认 L2。级别越高,AI 越自由(详见第七章)。
任务数
这个项目当前登记了多少任务。
累计花费
项目至今的累计花费金额,是红色高亮显示的。
1.3 "AI 预算消耗"卡:钱花到哪一步了
再往下是预算区。这里会显示一行文字:
当用量百分比达到预警线时,这里会出现一个琥珀色的「预警」标签,提醒你该考虑补充预算了。预警线由后端统一下发(默认 80%,卡片上会直接标出「预警线 N%」),和「计费明细」页是同一套口径,不会出现两个页面各说各话。
1.4 "预算运行态"卡:三道保险的实时状态
这一张卡片把三种"防烧钱保险"的状态并排显示:
| 标签 | 含义 |
|---|---|
| 熔断:是 / 否 | "是"表示预算已耗尽,循环被自动拉闸暂停 |
| 降级:是 / 否 | "是"表示系统正以降级模式运行(如模型/引擎降档以省成本) |
| 已终止:是 / 否 | "是"表示项目已进入终止态 |
卡片底部还会显示"总预算 ¥x / 已用 ¥y · AI ¥x / 已用 ¥y",把总预算和AI 运行预算两条线分开列清楚。
1.5 "项目已因兜底保护暂停"——最关键的一条报警
如果系统因为连续失败或预算问题自动刹车了,控制台顶部会出现一条醒目的告警,标题是:
原因:…… · 暂停时间:……
兜底暂停为持久状态(跨重启保留),需人工在运行配置 / 任务面板处理后,点击「恢复」继续。
兜底暂停是持久状态——就算你把项目服务器重启,它还是暂停的。这是故意的:出问题时必须由人去看一眼、处理掉根因,再手动点「恢复」。不处理就点恢复,很可能下一轮又立刻被刹停。
另外注意:处在这种状态时,顶部状态标签会显示「已暂停(兜底)」,不会再挂着绿色的「运行中」——别被一个绿标签骗过去,以为它还在正常干活。
1.6 十六个快捷入口
控制台下方排着一整屏快捷入口,它们是本章后面各节的入口,也是你日常最常点的位置(顺序如下):
任务管理 · 运行轮次 · 日志面板 · 计费明细 · 人工节点 · 角色管理 · 目标管理 · 审计治理 · 经营日报 · 监控指标 · 结项报告 · 验收记录 · 测试运行 · 阿米巴核算 · 经营驾驶舱 · 权限租赁
任务管理(我要 AI 干啥)、运行轮次(AI 现在干到哪了)、人工节点(有没有等我点确认的)、计费明细(花了多少钱)。其余入口用到再点,本章后面会逐个讲。
1.7 改运行模式:全自动 / 半自动 / 人工审核
点运行模式卡片旁的「修改」,会弹出「调整运行模式与预算科目」窗口。三个选项及其官方说明如下:
| 选项 | 界面上给你的说明(原文) |
|---|---|
| 全自动 | AI 自动拆解任务、调度轮次、评审验收,全程自动执行,仅在关键节点通知你。 |
| 半自动 | AI 自动执行,但在关键决策节点(目标变更、大额支出、对外动作等)由人工确认后继续。 |
| 人工审核 | AI 产出方案后必须人工审核通过才执行,节奏较慢但最可控。 |
选到「人工审核」时,界面上会出现一条提醒:
请记住:只有全自动和半自动模式会启用自动运营循环;切到「人工审核」后,循环会暂停,任务要靠你手动触发。另外,在创建项目向导里这个选项叫「手动」,进了项目控制台后叫「人工审核」,它们是同一个东西。
同一个窗口里还能调整"预算科目"(把 AI 的花费归到哪个科目)。界面提示:常用科目:token_fee(模型调用)/ third_party_api(第三方接口)/ compute_fee(算力)/ human_intervention(人工介入),留空科目将不计入。
二、任务:给工厂安排机床
工厂要开工,先得有活干。"任务"就是一件件要被 AI 完成的活。它是整个自动运营的基本单位——后面讲的时间片、轮次、验收、计费,全都围绕任务展开。
2.1 任务列表长什么样
进入「任务管理」,右上角有 新建任务。列表顶部有六个筛选标签,点一下就能只看某一类任务:待执行 / 运行中 / 已暂停 / 已完成 / 失败 / 规划中。
表格的列依次是:任务名称 / 状态 / 优先级 / 时间片 / 引擎 / 类型 / 模型 / 创建时间 / 操作。其中"模型"列如果没单独指定,会统一显示「路由自动」——意思是交给平台的模型网关自己挑合适的模型。
每一行的"操作"区最多会出现这几个按钮:编辑、继续规划(软件工程类处于规划中时)、继续修改(软件修改类处于规划中时)、查看规划(软件工程类已提交执行后,只读回看)、恢复(暂停时)、暂停(运行时)、删除(仅规划中)。
任务列表里,处于「规划中」的任务(也就是软件工程/软件修改建好但还没走完向导的那些)操作区会多出一个 删除 按钮,点了会先弹二次确认。这是给你清理"中途放弃的向导任务"用的。
反过来,已经进入待执行 / 运行中 / 已完成的任务不可删除——点了接口会返回 400 并说明原因。想让一个正在跑的任务不再执行,稳妥做法是暂停它,或编辑它的提示词模板把方向改掉,等下一次 review 重排。这样设计是为了防止误删正在推进或已验收留痕的任务。
2.2 新建任务时,每个字段怎么填
点 新建任务,弹窗里字段不少,但真正需要你想清楚的只有四五个。逐个说明:
| 字段 | 怎么理解 / 怎么填 |
|---|---|
| 任务名称(必填) | 一句话说清干什么,例如 placeholder 里给的示例:如:市场定向调研。别写"任务1"这种没信息量的名字。 |
| 描述(必填,最多 500 字) | 把要求写具体。特别重要:请把"什么样算做完"也写进这里(原因见 2.4)。 |
| 任务类型 | 三选一:通用任务 / 新建软件工程 / 软件修改。后两类会走软件工程专用流程(详见第 10 章)。 |
| 软件名称 | 只有"新建软件工程"才出现。留空则自动命名(按任务标题或序号)。填了它,这个软件的 PRD/TAD/模块文档就会写进独立的子目录,和项目里别的软件互不覆盖(详见第 10 章)。 |
| 优先级 | P0-紧急 / P1-高 / P2-常规 / P3-低。用来决定该任务在排班中的轻重。 |
| 时间片权重 | 1~10,默认 1。这是分配精力的旋钮:权重越高,每轮分给它的时间片越多。详见第三章。创建后不可修改。 |
| 引擎类型 | 循环执行(loop)适合复杂、编码、长时任务;Agent 智能体(Agent 引擎)适合信息整合、接口调用、快速任务。 |
| AI 模型 | 留空即「路由自动」,由网关按任务复杂度挑模型。 |
| 关联软件工程 | 仅"软件修改"类任务需要选。 |
| 时限(秒) | 默认 7200 秒(2 小时),步进 60。单轮超过这个时长会被强杀,防止无限运行。 |
| 角色 ID | 可选。placeholder:指派 Agent 角色 ID(可选)。指定后由这个 AI 员工来干。 |
| 提示词模板 | 可选。placeholder:任务执行提示词模板。想固定 AI 的干活套路时填。 |
在任务列表点「编辑」时,弹窗顶部会明确告诉你能改什么:可改——优先级、引擎类型、时限、AI 模型、提示词模板;不可改——任务名称、任务描述、时间片权重、角色 ID。
为什么把描述锁死?因为描述是独立验收 Agent 的对照依据(验收要拿"当初说好什么算做完"来判),中途改描述等于换了尺子。所以请一次就把"什么算做完"写清楚。补充或纠偏信息的正确出口是:编辑任务的描述(首次填写时)或任务级提示词模板——界面上没有独立的"注入信息"按钮,别找。
另外,编辑时「时限(秒)」留空表示保持原值,不会被悄悄重置成默认的 7200。
2.3 引擎怎么选:一个警示弹窗救了很多人
如果你选了"新建软件工程 / 软件修改"这类任务类型,却把引擎选成了 Agent 智能体,界面会弹出一条警告:
两条经验:要写代码、做工程、跑长任务的,选「循环执行」;只是查资料、做汇总、调接口的短活,选「Agent 智能体」。不指定时,系统会根据描述里的关键词自动猜(编码/开发/构建→循环;查询/汇总/快速→Agent;拿不准→循环)。引擎的最终优先级是:任务级 > 角色级 > 项目默认。
2.4 界面没有"验收标准"输入框,怎么办?
这是新手最容易踩的一个坑,务必看清:当前界面并没有一个独立的"验收标准"输入框(这个字段在系统接口层是存在的,只是暂时没有放到界面上)。所以,
这样做:把"什么算做完"直接写进任务描述里。例如:
产出 3 篇 B2B 英文邮件文案,每篇含主题行、正文、CTA 按钮文案,并通过事实自检。
别这样做:只写"写几篇营销文案"就提交。AI 不知道做到什么程度算达标,容易提前宣布完成,或反复返工。
写点营销文案。 ✗
判定任务"完成"的硬信号,是 AI 在输出末尾打出 `[Task finished]` 标记(详见第六章)。而它判断自己达没达标,依据就是你在描述里写的标准。所以,描述写得多清楚,AI 就干得多靠谱。
2.5 中途想补充信息怎么办
项目跑起来后,你常常会想补充需求,比如"客户要求周三前交付"。系统里"注入新信息"的说法确实存在,在你看到的那条空闲等待消息里也会出现。但要先明确一条规则:自动运营任务的「描述」创建后不可修改(它是独立验收的对照依据)。所以补充信息的可行路径是:
- 在任务列表找到那条任务,点 编辑;
- 把新信息写进任务级「提示词模板」(不要试图改描述,编辑态下它是只读的);
- 保存。下一轮调度到它时,AI 就会看到更新后的提示词。
如果改动大到连目标都变了,更干净的做法是新建一个任务,让旧任务走完或被暂停。
另外,如果你用的是"智能体"里的 Agent 任务(第 08 章),那个页面有一个专门的 注入 按钮,可以在任务运行中实时投喂信息。两者不要混淆:自动运营任务靠"编辑描述",Agent 任务靠"注入信息"。
三、时间片与轮次:排班表怎么转起来
这是本章最"硬核"的一节,但只要抓住一个比喻就好懂:排班表上有 10 个格子(时间片),工人每上一班(一轮)就照表做一个格子的活。
3.1 10 个时间片,任务按权重"占格子"
系统默认把调度表切成 10 个时间片。每个任务按它的时间片权重(1~10)去"占格子":
- 权重 1 的任务:占 1 个格子,每 10 轮才轮到它一次
- 权重 3 的任务:占 3 个格子,出现频率是权重 1 的三倍
- 权重 10 的任务:占满全部格子,几乎每轮都在干
所以"时间片权重"本质上是你给它分配的精力比例。重要的、要尽快出结果的活,权重调高;日常维护类的小活,权重给 1 就行。
如果未完成任务的权重加起来超过了 10,系统会自动把格子扩到够用,保证没有任务会被"漏掉"。你不需要手动算格子数。
3.2 一轮 = 一个格子的活
每推进一个时间片,就产生一次轮次(round)。轮次是整个自动运营的"心跳"。轮到某个任务时,系统会:
- 把它上一轮留下的任务接力信息注入提示词(见 3.3);
- 调用引擎真的去干活(跑代码、调模型、调接口);
- 把这一轮的执行记录、耗时、花费、日志都落下来;
- 判断这一轮的产出是否出现了完成标记。
轮次分三种模式,你在「运行轮次」页面的"模式"列能看到:
| 模式 | 叫什么 | 干什么 |
|---|---|---|
| task | 任务轮 | 按排班表挑一个未完成任务,干一个时间片的活 |
| review | review 轮 | 让 AI 抬头看全局,重排任务与时间片(见第四章) |
| free | 空闲等待轮 | 没活可干时待工省电,只做常规检查(见第五章) |
3.3 任务接力:AI 为什么能"接着上一轮继续干"
这是很多新手最好奇的点:AI 又没有记忆,凭什么下一轮能接着上轮干?答案是——每轮结束时,系统会让它写一张"交接条",内容包括:
- 本轮目标是什么;
- 实际做了哪些动作;
- 还有什么没做完;
- 下一步该干什么。
这张交接条会保存下来,下一轮轮到同一个任务时,自动注入提示词。AI 就像工人翻开上一班的交接本,照着"下一步"接着干。这个机制,读起来像是"接力棒",所以本手册统一叫它任务接力。
接力信息记录的是进度(干到哪、下一步干啥),不是验收结论。任务的最终结论由独立验收 Agent 给出(第六章)。这也是为什么"完成"必须靠硬标记——光靠接力说"快好了"是不算数的。
3.4 怎么看 AI 干到哪了:运行轮次页
页面标题是「运行轮次与日志」,表格列有:轮次 / 状态 / 模式 / 引擎 / 耗时(秒)/ 花费(元)/ 开始时间。你可以一眼看到每一轮干得好不好、花了多少钱。
"状态"列的取值有:待执行 / 运行中 / 已通过 / 需重做 / 已驳回 / 失败。后三个(需重做、已驳回、失败)出现时就要留意了,说明这一轮没过关或出了问题。
点开任意一轮,可以看它的实时日志:
如果实时连接断了,日志面板会显示一个标签「实时连接已断开,使用轮询」,然后自动改用轮询刷新——不影响你看日志,只是刷新没那么"丝滑"。
3.5 单轮时限:2 小时的"熔断保险丝"
每个任务有一个"时限"字段,默认 7200 秒(2 小时)。这是单轮执行的兜底:万一 AI 卡进死循环或某个外部接口一直不返回,超过时限进程会被强制结束,不会让一轮无限跑下去、把钱和时间都烧光。
你可以按任务复杂度调整它:简单的信息汇总给个 600~1800 秒就够;跑大型代码构建的,给到 7200 秒甚至更长。
3.6 日志面板:想看某次执行到底聊了啥
如果说"运行轮次"是总览,那"日志面板"就是放大镜。它的表格列有:任务 / 轮次 / 状态 / 日志文件 / 更新时间。状态只有两种:运行中(对应正在执行的)和已结束。如果还没有任何日志,空态会提示「暂无日志绑定(任务开始执行后自动生成)」。
点开某一条,就能看这次执行的完整对话记录,面板标题是:
日志会按"项目 → 任务 → 轮次"的顺序组织,你可以顺着往下钻,看 AI 每一步在想什么、调了什么工具、拿到了什么结果。日志支持实时推送和断线重连,刷新是自动的——你不用手动狂点刷新键。
当某个任务反复失败、或验收总是不通过时,最有用的动作不是反复重启,而是打开日志面板,看 AI 最后一次执行卡在哪一步。多半能一眼看出是"外部接口挂了"还是"任务本身描述有歧义"。
四、review 轮:让 AI 抬头看全局,重排任务
如果工厂只会闷头干表上排好的活,早晚会出问题:环境变了、客户需求变了、某件事其实早该停了……所以这套机制安排了一个"定期复盘"的动作,叫 review 轮。
4.1 什么时候会自动触发 review
满足下面任意一条,系统就会插入一轮 review:
| 触发条件 | 说明 |
|---|---|
| 间隔触发 | 距上次 review 已经过了 20 轮(默认值,可配置) |
| 全完成强制触发 | 所有任务都已完成,强制做一次 review 决定下一步 |
| 手动触发 | 你主动要求立刻重排(见 4.3) |
注意:如果项目正处在"空闲等待"模式(没有未完成任务),系统会忽略"全完成"这条触发,避免陷入"空转→review→还是空→再 review"的死循环。
4.2 review 轮里 AI 到底在看什么
到点后,AI 会"抬头"审视全局,看的东西包括:
- 当前所有任务的进度与完成情况
- 代码/文件的变更(判断有没有实质性推进)
- 预算的消耗速度(钱还够不够)
- 收益与产出(做出来的东西有没有价值)
然后,它会产出一份"新的排班方案"——重新排布任务集和它们占用的时间片。这份方案会被系统校验后才生效;校验不通过就丢弃重来,不会把乱掉的排班写进去。
4.3 手动触发 review
大多数情况下,AI 会按节奏自动 review。但有时你刚补了需求、或想立刻重排,就可以主动触发一次。
在运行轮次页和自动运营控制台上,都补上了「触发 review」按钮:点一下,系统会在当前轮跑完后插入一次 review 重排。项目里的 AI 对话同样有效(用自然语言说"帮我重排一下任务"),两条路都通。这也对上了第 2.5 节那条空闲等待消息里提示的"触发 review 重排任务"。以实际界面为准。
4.4 review 也会失败,而且有兜底
review 轮本身也可能失败(比如 AI 输出的方案格式不对、模型调用出错)。系统会记一个"review 连续失败计数",处理方式和任务失败一样:连续失败达上限(默认 3 次)就告警并暂停项目循环,等人工介入。这是防烧钱的一环,不要把它当成 bug。
失败计数是连续计数:只要有一次 review 成功,之前的失败记录就归零了。所以偶发的失败不会累积成"误熔断"。
五、空闲等待(free):没活干时,别空转烧钱
工厂没订单时,聪明的做法是关灯待工,而不是让机器空转。这套机制也是这样——当没有未完成任务(任务都完成了,或任务集为空)时,项目进入空闲等待模式。
5.1 进入空闲等待后会看到什么
此时系统只做常规检查,不再每一轮都调用 AI。当空闲累计到一定轮数,你会收到一条通知,原文是:
在「运行轮次」页,你能看到这些轮次的模式显示为 free。
5.2 "不再消耗 LLM"是什么意思
意思是:空闲等待期间,系统不会逐轮去调模型,因此几乎不产生 token 费用。这对新手特别友好——任务做完了忘了管,也不会默默地一直烧钱。
空闲累计到 10 轮、20 轮、30 轮……这些节点时,系统会尝试让 AI 自己拆解出一批新任务(这叫"AI 补货")。成功拆出新任务,项目就自动退出空闲、继续开工;没拆出来,就继续待工、下个节点再试。所以"空闲"不等于项目死了,只是它暂时没活干。
5.3 怎么把项目从空闲状态"唤醒"
通知里其实已经把答案告诉你了,两步:
- 注入新信息:在「任务管理」里新建任务,或编辑已有任务补充新要求(见 2.5);
- 触发 review 重排:让 AI 重新看一遍任务集,规划出未完成任务,从而退出空闲模式。
光加任务有时还不够——项目的 free 状态是"按任务集重算"的,需要有未完成任务才能退出。最稳的组合是:补任务 + 让它重排一次。如果补了任务后长时间还没动静,就主动触发一次 review。
六、验收:三权分立,谁也不能自审自批
AI 说"我干完了",到底能不能算数?这套机制给出的答案很硬核:不能自审自批。干活的一拨、验收的一拨、批准的一拨,三方分开,这就是三权分立验收。
6.1 一次验收的完整流程
[Task finished]
对照标准评审
(标完成)
(重做)
(升级人工)
验收 Agent 的角色,是独立于执行者的——同一件事不会由干活的 AI 自己打分。它评审的依据,就是你写进任务描述里的"什么算做完"。
6.2 验收的三种结论
| 结论 | 英文 | 含义与后果 |
|---|---|---|
| 通过 | pass | 认定达到标准,任务标记为完成 |
| 返工 | redo | 没达标,退回让 AI 重做(会累计返工次数) |
| 驳回 | reject | 问题较严重,升级到人工处理 |
返工和驳回都不会无限循环:系统对"驳回"设有上限(默认 3 次),达到阈值就升级人工,防止 AI 在一件事上反复重跑、猛烧钱。
6.3 验收记录页:每一笔验收都留痕
页面标题「验收记录」,顶部可按验收结论(通过 / 返工 / 驳回)、人工状态(待审批 / 已批准 / 已拒绝)、以及任务 ID筛选。
表格列有:验收 ID / 任务 / 结论 / 评分 / 报告 / 人工状态 / 抽样 / 成本 / 时间 / 操作。点「详情」会打开「验收详情」窗口,里面有:验收 ID、任务 ID、执行者、验收 Agent、结论、评分、人工状态、是否抽样、Token 输入、Token 输出、成本,以及三块正文——验收报告、理由(reasons)、证据(evidence_paths)。
这正是三权分立的体现:你可以清楚地看到"这活是谁干的"和"这活是谁验的"。如果两个字段指向同一个角色,那就不符合三权分立原则了——不过正常情况下系统会保证它们是分开的。
「抽样」这一列也值得注意:不是每一份产出都会被人工复核,系统会按比例抽样,被抽中的会进入人工审批流程,人工状态随之变为"已批准 / 已拒绝"。
七、人工处理节点:需要你点头的地方
不是所有事都能让 AI 自己拍板。涉及合规风险、花钱、对外发布、删除数据的动作,必须有人参与。这套机制把这些"等人点头"的环节统一成一种东西——人工处理节点。
7.1 三种通道:红黄绿
每个节点都会被系统打上一个"通道"标签,代表它的敏感程度:
绿-例行
例行事项。按自主级别处理,L0 直接执行归档,一般不需要你操心。
黄-敏感
敏感写操作(发布、删除、付费、外发等)。会生成"权限租赁",超权限上限需授权。
红-强制
命中红通道禁止清单。强制 L3 人工审核,AI 不得代行。
7.2 自主级别 L0~L3:AI 能自主到哪一步
项目有一个"自主级别"(默认 L2),它决定了 AI 遇到需要决策的节点时,是"自己干"还是"等你点"。级别从低到高:
| 级别 | 行为 | 给新手的建议 |
|---|---|---|
| L0 | 全自主执行,不创建节点、也不通知你 | 只在你非常信任这类事时才用 |
| L1 | 通知不等待:创建节点+通知你,但 AI 继续推进 | 想"知会一声"又不阻塞进度时用 |
| L2(默认) | 一键确认:AI 暂停等待,你在面板点一下确认才继续 | 推荐。平衡了效率与安全 |
| L3 | 强制人工审核:必须审核通过才继续 | 高风险、合规相关的活 |
这套级别还有一层"聪明"的地方:系统会按 AI 的历史表现给一个"渐进信任分",分数高就允许更自主(往 L0 靠),分数低就收得更紧(往 L3 靠)。干得好,权限自然放开;干得差,权限自动收紧。
7.3 人工节点页长什么样
页面标题「人工处理节点」,右上角有 新建节点。顶部筛选标签:待处理 / 处理中 / 已完成 / 已驳回 / 已升级。
每个节点以卡片展示,卡片上有:通道、自主级别(L…)、SLA(秒)、处理人、描述。可用的操作按钮是:
| 按钮 | 作用 |
|---|---|
| 确认完成 | 批准这个节点,AI 继续 |
| 通知催促 | 重新发一次通知(界面会提示"节点已确认完成/已发送通知"等结果) |
| 升级处理 | 把节点往上抬一级,交给更上级处理 |
| 移动审批 | 跳到移动审批页面去处理 |
7.4 手动建一个节点时填什么
点「新建节点」,弹窗的字段有:标题(必填,如 如:审核营销文案)、描述、自主级别(L0-全自主执行 / L1-通知不等待 / L2-一键确认 / L3-强制人工审核)、关联任务 ID(可选)、SLA 超时(秒)(默认 86400,步进 3600)。
你会发现新建表单里没有"通道"这个字段——因为通道是系统根据动作敏感度自动判定的,你只需要在显示时看它是什么颜色就行,不需要(也不能)手动指定。
7.5 SLA 与双签:节点也会"超时"和"双重把关"
每个节点都有一个 SLA(处理时限)。超过时限没处理,系统会有两种处理方式:配置了"超时降级"的,就降为 L1"通知不等待"、让循环继续;没配置的,就按"升级链"逐级往上找负责人(项目负责人 → 平台超管)。升级链也用尽时,节点会保持挂起——它不会自动放行敏感动作,只是安静地等着人。
对高风险节点(合规、红通道),系统默认要求双签复核(也就是"四眼原则"):需要两位不同的复核人依次确认。第一位确认后节点仍是待处理状态,会去通知第二位;两位都批了才算完成。同一个人没法"双签",任一复核人拒绝,节点即被驳回。
7.6 权限租赁:临时的"放行条"
黄通道的敏感动作,可以申请一张临时的"放行条",即权限租赁。它绑定三样东西:动作(做什么)、到期时间(有效到什么时候)、成本上限(最多花多少钱)。到期或花钱超限就自动回收;执行前系统会检查这张条子还有没有效。
控制台里有一个 权限租赁 快捷入口,可以查看和吊销这些放行条。
八、失败与中断:出问题时,系统怎么刹车
再好的工厂也会出故障。区别在于:好的系统出问题时能安全地停下来,而不是一路烧钱到天亮。这一节讲三道刹车。
8.1 第一道刹车:连续失败的三级兜底
同一个任务连续失败时,系统不是简单地重试,而是逐级加码:
降级重试
升级人工
告警退出
| 阶段 | 系统做什么 |
|---|---|
| 第 1~2 次(降级重试) | 依次尝试:换引擎 → 换角色版本 → 缩小任务范围。换个思路再试,多半能救回来。 |
| 第 3 次(升级) | 让管理者 AI 复盘,并创建一个人工处理节点通知负责人——该人来拿主意了。 |
| 超过上限(默认 3 次) | 告警退出:发通知 + 暂停项目循环,彻底停手防烧钱。 |
这里的降级指的是换策略(换个引擎、换个角色版本、把任务范围缩小一点),目的是绕开当前失败的路径,让任务能继续推进,而不是降低质量标准。
8.2 第二道刹车:预算预警与熔断
钱是最硬的约束。系统对预算设了两道线:
- 预警线(默认 80%):达到时发预算预警通知,提醒你快到上限了;
- 熔断线(超预算):AI 运行预算或总预算任一超限,就暂停循环,并通知"预算耗尽,请补充预算后继续";
- 单轮上限(默认 100 元/轮):每个任务可以设一个"单轮最大预算"。轮末结算时如果这一轮实际花费超过这个上限,系统会告警并暂停项目,防止某一轮"一口气烧掉一大笔"。这是最后一道按"单班"计的保险,和上面按"总额"计的两条线不冲突。
补充预算后,在控制台点「恢复」或「启动」即可继续——系统会自动复核两条预算线并清除熔断标记。
如果预算仍然超限,「恢复」会被拒绝(提示"预算已耗尽,请补充预算后继续")。正确的顺序是:先补充预算,再点恢复。
8.3 紧急停止:KillSwitch
万一出现你完全无法控制的情况(比如 AI 正在执行明显危险的动作),系统提供"紧急停止"开关。它的效果等价于「停止」——硬停循环、状态置为已停止。这是一个"红色按钮",用于最极端的情况。
8.4 中断恢复:断了之后怎么接上
项目可能因为各种原因中断:你点了暂停、人工节点超时、预算熔断、服务器重启……恢复时,系统会按"断了多久"区别对待:
| 中断时长 | 系统怎么做 |
|---|---|
| 豁免期内(默认 2 天内) | 不做 AI 评估,直接"干净续接"——环境大概率没变,接着干就行 |
| 超过豁免期 | 先做环境漂移检查(代码有没有改、依赖有没有变、凭据有没有失效、数据库结构有没有动、知识库有没有更新) |
漂移检查之后,系统按中断时长分级(小于 7 天 / 7~30 天 / 超过 30 天),给出三种结论之一:
- resume(直接续接):环境没实质变化,接着原来的干
- resume_with_adjust(调整后续接):环境有变化,微调方案后继续
- replan(重新规划):变化太大,重排任务再开始
这些评估结论和最终的人工决定都会留痕,方便你日后回看"当时为什么这么处理"。
想象你出差两周回来,桌上那份工作计划的背景可能已经变了:客户换了需求、代码被别人改过、某个 API Key 过期了。中断越久,这些"环境漂移"的概率越高,所以系统要先检查、再决定是"照旧干"还是"重新规划"。
8.5 收尾:终止项目与结项报告
当项目真正做完(或你决定不再做了),点控制台的 终止项目 并填写原因,系统会置为终止态,并自动生成一份结项报告。你也可以随时通过 结项报告 快捷入口查看最近一份。
结项报告通常包含五块内容:目标达成情况、任务完成与返工率、花费与收益、知识沉淀、经验总结。它是做阶段性复盘、或向投资人/老板汇报项目成果时最好用的一份材料。
终止之后项目就进入终态了,不会再有新的自动运营轮次。所以点它之前,先确认"这个项目确实告一段落了"。如果只是想让它歇一歇,用「暂停」或「停止」,不要用「终止」。
另外还有一个 测试运行 入口,用来查看任务的自检式测试记录(测试 ID、任务、是否通过、引擎、改动说明、测试目标、耗时、时间,以及详情里的"输出尾部""错误信息")。它适合在开发类项目里快速确认"这次改动测过了没有"。
九、计费明细:每一分钱花在哪
自动运营跑起来,钱就像水一样在流。这一页让你把水表看清楚。
9.1 四张汇总卡
累计花费
红色大数字,项目至今花了多少钱。
预算已用
AI 运行预算里已经用掉多少。
输入 Token
累计喂给模型的 token 数量。
输出 Token
累计模型生成的 token 数量。
9.2 计费单价:钱是这么算出来的
AI 的花费,本质上是 token 用量乘以单价。默认单价如下(可在运行配置里调整):
| 类型 | 默认单价 | 说明 |
|---|---|---|
| 普通输入 | 1 元 / 百万 token | 含缓存创建部分,统一归入输入 |
| 输出 | 2 元 / 百万 token | 模型生成的部分 |
| 缓存读 | 0.02 元 / 百万 token | 命中缓存的读取,便宜很多 |
举个例子:输入 100 万 token、输出 50 万 token、缓存读 1000 万 token,总费用约 2.2 元(1×1 + 0.5×2 + 10×0.02)。
有个细节对财务很重要:单价改了,历史流水不会重算。每一笔开销在发生时就按当时的单价"定格"了,后面的调价不影响已经记好的账。
9.3 那两个标签一定要看懂:估算 / 未计量
在"累计花费"卡片旁边,你可能会看到两个小标签。它们是理解这份账单"靠不靠谱"的关键,请务必看清它们各自的官方解释:
"含估算"的部分是按文本长度估出来的,上游没返回用量时才会产生;"未计量"的轮次真的执行了但没读到用量,只按 0 元留痕。所以:不要把这里的数字直接拿去对账或核销。精确账单以平台账本为准。
9.4 按角色、按天看分布
页面下方有两张表,帮你回答"钱被谁花了、哪天花得最多":
- 按角色花费分布:列有「角色 / 花费(元)/ 其中估算(元)」。这就是"岗位级核算"的基础——你能看到哪个 AI 员工最费钱,从而优化它的提示词或换更省的模型。
- 按天花费分布:列有「日期 / 输入 Token / 输出 Token / 花费(元)/ 其中估算(元)」。突然某天花得特别多,多半是那天在跑一个新任务或一个复杂构建。
页面顶部还有一个"预算消耗"进度条,显示「预算 ¥x / 已用 ¥y」,并用颜色和「已熔断 / 预警」标签提示状态。
十、目标管理:让 AI 干活盯着"目标",而不是"任务清单"
任务是一条条"活",但如果 AI 只盯着任务清单,很容易跑偏——做了一堆活,却没朝你真正想要的方向走。为了解决这个问题,系统引入了一层更高的东西:目标树。
10.1 目标树:愿景 → 目标 → 关键结果 → 任务
它是一棵层级树:最顶层是你的愿景,往下拆成一个个目标,每个目标再拆成若干关键结果(KR),KR 最终挂到具体任务上。这样,每一个任务都知道自己"为了什么"而做。
页面标题「目标管理」,右上角 新建目标。列表里目标的状态有三种:进行中 / 已达成 / 已归档。
10.2 一个目标里都有什么
点开一个目标,能看到:
| 区块 | 内容 |
|---|---|
| 关键结果(KR) | 每个 KR 有「KR 名称 / 指标 / 目标值 / 当前值」。达成率按各 KR 的权重加权计算。 |
| 关联任务 | 这个目标/ KR 下挂着哪些任务(空态显示"暂未关联任务") |
| 权衡权重 | 四项:成本 / 质量 / 风险 / 速度。四项归一化后相加为 1,不填时默认等权(各 0.25)。 |
| 升级阈值 | KR 的加权达成率低于这个阈值时,触发 review 或人工确认。 |
| 父目标 | 它在树上的上一级(顶级目标没有父目标)。 |
10.3 权衡权重:告诉 AI"你更在乎什么"
这四项权重非常实用,是新手最该用起来的一个能力。举个例子:
赶进度的项目:速度 0.4 质量 0.3 成本 0.2 风险 0.1
AI 会更倾向于快速出结果,容忍一定的试错成本。
合规敏感的项目:应把风险的权重调高、成本压低。
如果权重全填成默认等权,AI 可能会为了省钱而承担你不愿承担的风险。
换算成"人话":权重就是你的偏好票。你投给哪一项的权重高,AI 在做取舍时就往那个方向偏。
目标的创建、KR、权重、阈值这些配置和展示是能用的;但"AI 自动把任务拆到 KR 上""任务完成自动回填 KR 进度"这类联动,目前还在推进中。所以现阶段,目标树更多是给你和 AI 一个"共同的靶子",还需要人来对齐。以实际界面为准。
10.4 用对话来管目标
你还可以不点按钮,直接用自然语言在项目对话里驱动管理动作,例如:"帮我新建一个目标:本季度海外询盘量增长 30%""看看现在的目标都达成得怎么样了""把"市场调研"任务的优先级调高一点"。系统内置了一组管理工具,能理解这类指令并落到对应的操作上。写操作(删除、改预算、终止、对外发布)默认会要求人工确认,不会悄悄执行。
十一、日常操作节奏:每天、每周、每月该干什么
机制都懂了,最后落到"你每天实际要动手多久"。给你一份可照做的节奏表。
11.1 每天(5~10 分钟)
- 打开自动运营控制台,确认状态是「运行中」,没有出现"兜底保护暂停"告警
- 扫一眼人工节点:有没有"待处理"的等着你点「确认完成」
- 扫一眼运行轮次:有没有"需重做 / 已驳回 / 失败"的轮次
- 看一眼累计花费:涨得是不是符合预期
11.2 每周(20~30 分钟)
- 看计费明细的"按角色分布"和"按天分布",找出最费钱的角色和日子
- 看验收记录:返工和驳回多不多?多的话,回头把"什么算做完"写得更清楚
- 看目标管理:KR 的达成率有没有在往好的方向走
- 该补的任务补进去,该调的权重调一调,然后触发一次 review 重排
11.3 每月(1~2 小时)
- 看审计治理 / 经营日报 / 结项报告,做一次阶段性复盘
- 根据实际花费,重新评估 AI 运行预算够不够、要不要调单价
- 清理长期不动的任务,或归档已完成的,保持排班表干净
不是"看数字",而是把任务描述写好。你会发现,凡是返工多、花费高的项目,十有八九是任务描述写得含糊。花十分钟把"什么算做完"写清楚,能省下后面几十上百轮的返工和 token 花费。
11.4 新手最常见的五个误区
误区一:一条大指令干所有事。
把"帮我做营销、发邮件、找客户"塞进一个任务,AI 会不知道从哪下手,验收也没法评。正确做法:拆成"市场调研""写 3 封开发信""发送并跟进"等独立任务。
正解:一个任务对应一件可验收的产出物。
每件产出的"什么算做完"都能一句话说清,验收才有依据。
误区二:所有任务都给高优先级、高权重。
结果就是"人人都是重点=没有重点",紧急的活被摊平,反而更慢。
正解:P0 和高权重留给 1~2 件真正要紧的活。
其余保持 P2、权重 1,让排班表有层次。
误区三:项目卡住了就反复"恢复/启动"。
如果是兜底保护暂停,根因没处理,点了恢复下一轮又被刹停,白折腾。
正解:先看告警原因和日志,处理根因,再恢复。
控制台告警和日志面板,就是给你排查用的。
误区四:把"自动运营"当成"不用管"。
人工节点、验收抽样、预算预警,都需要你定期花几分钟。完全不管,项目迟早卡在某个等你点头的节点上。
正解:每天 5 分钟看一眼,胜过一周后救火。
按 11.1 的四项清单扫一遍即可。
误区五:把计费明细当成精确账单。
里面含"估算"和"未计量"部分,直接拿去对账会出错。
正解:计费明细用来看趋势、做优化,精确账单看平台账本。
两者口径不同,各司其职。
11.5 让 AI 帮你管项目
最后分享一个进阶技巧:这套系统里,很多管理动作都可以用自然语言驱动。你可以在项目对话里直接说,例如:
把"市场调研"任务的优先级调到 P0,权重调到 3。
帮我触发一次 review,重新排一下任务。
最近一周 AI 花了多少钱?哪个角色花得最多?
有哪些人工节点在等我处理?
系统读到这类指令,会自动落到对应的管理操作上。涉及删除、改预算、终止、对外发布等重大写操作时,默认会先要求你确认,不会擅自执行。
十二、本章小结与下一步
这一章内容很密,我们用一句话把整套机制串起来:给工厂排好班(任务+时间片),让它一轮一轮干(轮次+接力),定期抬头重排(review),没活就待工(空闲等待),干完交给独立质检(验收),遇事等人点头(人工节点),出问题就刹车(兜底+预算熔断),全程记好账(计费)。
核心要点回顾
- 控制台是总控室:启动 / 暂停 / 恢复 / 停止 / 终止,四个状态搞清楚;"兜底保护暂停"是持久状态,必须人工处理后手动恢复。
- 任务的基本单位是"活":写清描述、写好"什么算做完";权重决定精力分配;要交付软件就用"循环执行"。
- 10 个时间片 + 任务接力 = 排班表:每轮干一个格子的活,轮末写交接条,下轮接着干。
- review 轮定期重排(默认 20 轮或全完成触发);空闲等待不烧钱,靠"注入新信息 + 触发 review"唤醒。
- 验收三权分立:完成靠 `[Task finished]` 标记触发独立验收,结论分通过 / 返工 / 驳回。
- 三道刹车:连续失败三级兜底、预算 80% 预警与超限熔断、紧急停止开关。
- 计费是运营参考而非发票:看懂"估算 / 未计量"两个标签。
下一步
到这里,你已经能独立地把一个项目"跑起来"并"管起来"了。但项目里那些真正复杂的活——比如开发一个新功能、修改一个已有的软件工程——还有一套专门的正道。下一章我们讲:
你会看到"软件工程向导"的七个步骤、"软件修改"弹窗怎么用,以及如何用"新建任务"这个正确姿势给项目加功能。
附录 A · 任务描述模板全集
下面 14 条模板,覆盖了新手最常遇到的任务类型。用法:用方括号里的内容替换成你的项目实际信息,直接粘进「任务描述」。每条都包含"什么算做完",这正是 AI 判断是否达标的依据。
附录 B · 状态与术语全表
B-1 任务状态
| 值 | 界面中文 | 含义 |
|---|---|---|
| pending | 待执行 | 已登记,等排班轮到它 |
| running | 运行中 | 正在执行中 |
| paused | 已暂停 | 被手动暂停,不再被调度 |
| done | 已完成 | 验收通过 |
| failed | 失败 | 执行失败,进入兜底流程 |
| planning | 规划中 | 软件工程/软件修改类任务还在前期规划 |
B-2 轮次状态
| 值 | 界面中文 |
|---|---|
| pending | 待执行 |
| running | 运行中 |
| passed | 已通过 |
| redo | 需重做 |
| rejected | 已驳回 |
| failed | 失败 |
B-3 轮次模式
| 值 | 中文 | 在干什么 |
|---|---|---|
| task | 任务轮 | 正常干一个时间片的活 |
| review | review 轮 | 重排任务与时间片 |
| free | 空闲等待轮 | 没活干,待工省电 |
B-4 验收结论 / 人工状态
| 类别 | 值 → 中文 |
|---|---|
| 验收结论 | pass → 通过;redo → 返工;reject → 驳回 |
| 人工状态 | pending → 待审批;approved → 已批准;rejected → 已拒绝 |
| 人工节点 | 待处理 / 处理中 / 已完成 / 已驳回 / 已升级 |
| 通道 | red → 红-强制;yellow → 黄-敏感;green → 绿-例行 |
| 自主级别 | L0 全自主 / L1 通知不等待 / L2 一键确认 / L3 强制人工审核 |
| 运行模式 | full_auto → 全自动;semi_auto → 半自动;manual_review → 人工审核 |
| 目标状态 | 进行中 / 已达成 / 已归档 |
| 引擎 | loop → 循环执行;agent → Agent 智能体 |
| 任务类型 | general → 通用;eng → 软件工程;mod → 软件修改 |
B-5 术语人话对照
| 你可能会听到 | 人话解释 |
|---|---|
| 自动运营 / auto-ops | AI 自己排班干活的那套机制 |
| 轮次 / round | AI 的"一上班",一轮处理一个时间片的活 |
| 时间片 / 时间片权重 | 排班表上的格子;权重决定这个任务每轮能占几个格子(精力比例) |
| 任务接力 | 每轮末写一张交接条,下轮接着干 |
| review 轮 | 让 AI 抬头看全局、重排任务 |
| 空闲等待 / free | 没活干时待工省电,不逐轮烧 token |
| 三权分立验收 | 干活的、验收的、批准的不是同一个 AI |
| 人工处理节点 | 需要你点一下才能继续的节点 |
| 三通道 red/yellow/green | 强制人工 / 敏感需确认 / 例行通知 |
| 自主级别 L0–L3 | 越高级别 AI 越自由,L2 是默认(需一键确认) |
| 渐进式信任 | 按 AI 的历史表现逐步放开或收紧权限 |
| 兜底保护 | 出异常时自动刹车防烧钱的保险 |
| 熔断 | 预算超限,循环被自动暂停 |
| KillSwitch | 紧急停止的红色按钮 |
| 权限租赁 | 给敏感动作开的临时"放行条",绑定动作、到期时间、成本上限 |
| 环境漂移 | 中断期间代码/依赖/凭据/数据库/知识库发生的变化 |
附录 C · 排班调度 20 问
1. 我的项目启动了但一直没动静,怎么排查?
按顺序查三件事:①运行模式是不是「全自动」或「半自动」("人工审核"不会自动跑);②自动运营是否已启用;③控制台有没有"兜底保护暂停"告警。三者都正常,再看「任务管理」里有没有任务——没有任务自然没活干。
2. 什么是"时间片"?我要自己去分配吗?
时间片就是排班表上的 10 个格子,系统自动分配,你不用手动排。你要做的只是给任务设"时间片权重"(1~10),决定它占几个格子。权重越高,轮到它的频率越高。
3. 权重设 10 会怎样?会不会把别的任务饿死?
权重 10 的任务几乎每轮都在跑,其它任务的轮次会明显减少。所以别给所有任务都设高权重——那样等于没设。把高权重留给真正紧急重要的 1~2 件活。
4. 任务多了会不会有任务永远轮不到?
不会。未完成任务的权重总和超过 10 时,系统会自动扩容时间片,保证每个任务都能被排上。
5. AI 说干完了,但我觉得没做完,怎么办?
多半是"什么算做完"没写清楚。把任务描述改具体(参考附录 A 的模板),然后触发一次 review 重排。系统也有独立验收 Agent 会把关,验收不通过会退回返工。
6. `[Task finished]` 是什么?我能自己写吗?
它是 AI 在输出末尾打出的"完成标记",系统检测到它才会触发验收。你不需要(也不该)手写它——它是给系统看的信号。你要做的是把"达标标准"写进描述,让 AI 判断何时该打这个标记。
7. review 轮什么时候来?我能要求它立刻来吗?
默认每 20 轮来一次,或所有任务完成时强制来一次。想立刻来,点运行轮次页或自动运营控制台上的「触发 review」按钮即可;在项目对话里说"帮我重排一下任务"同样有效。
8. AI 会不会把我不想删的任务删掉?
review 重排时 AI 确实会重新给出任务集。为了安全,系统会对它产出的排班做校验,不合规的取值会被纠正或丢弃重来。但"少列出一个任务"这种做法,本质上是把该任务移出排班——如果你发现重要的任务莫名消失了,把描述写得更明确、或给它固定更高的权重,并从「任务管理」重新添加。
9. 项目一直在"空闲等待",怎么让它继续干活?
两步:①注入新信息(新建任务或编辑任务补充要求);②触发一次 review 重排。只加任务不重排,有时它还在待工。
10. 空闲等待会一直烧钱吗?
不会。空闲期间不逐轮调模型,通知原文就写着"不再消耗 LLM"。它只在每 10 轮这些节点上尝试"AI 补货"拆新任务,频率很低。
11. 暂停和停止有什么区别?我该用哪个?
暂停是"歇一会儿",当前轮跑完进入等待,随时能「恢复」;停止是"收工",连服务重启都不自动拉起。临时改动用暂停,长期不跑用停止。
12. 为什么暂停后当前这一步还在跑?
这是故意的。暂停不会强杀正在执行的子进程,避免丢掉它已经积累的上下文。等这一轮自然结束,它才进入等待。
13. 项目因为"兜底保护"暂停了,点恢复为什么没用?
兜底暂停是持久状态,光点恢复可能下一轮又被刹停。正确做法:先去"运行配置 / 任务面板"处理掉触发兜底的原因(连续失败、预算超限等),再点「恢复」。注意此时顶部状态标签显示的是「已暂停(兜底)」,不要看到它还挂着"运行中"就以为没事。
14. 连续失败几次会停?
同一任务第 1~2 次失败会降级重试(换引擎→换角色版本→缩小范围),第 3 次升级到人工,超过上限(默认 3 次)就告警并暂停循环。review 轮连续失败同理。
15. 预算到多少会预警?超了会怎样?
默认在 80% 预警;超预算就熔断暂停,并通知你补充预算。补完钱后在控制台点「恢复」或「启动」即可,系统会自动清熔断标记。
16. 中断很久之后再恢复,会不会接不上?
豁免期(默认 2 天)内是"干净续接";超过豁免期,系统会先做环境漂移检查、按时长分级,给出"直接续接 / 调整后续接 / 重新规划"三种结论之一。
17. 计费明细里的钱和实际账单对得上吗?
不一定完全对得上。里面有"按文本长度估算"的兜底部分和"未计量"的轮次,所以这一页是运营参考,不要当发票核销。精确账单以平台账本为准。
18. 单价改了,之前的花费会重算吗?
不会。每笔开销在发生时按当时单价"定格",后续调价不追溯历史。
19. 我点了"人工审核"模式,任务为什么不动了?
因为"人工审核"不启用自动运营循环,任务需要你手动审核/触发才执行。想让它自动跑,切回"全自动"或"半自动"。
20. 目标管理里的"权衡权重"怎么填才对?
四项相加为 1,按你在乎的程度分配。不填时默认等权(各 0.25)。赶进度就抬"速度",重合规就抬"风险",控成本就抬"成本"。它决定了 AI 遇到取舍时往哪边偏。
附录 D · 成本优化清单(15 条)
- 把"什么算做完"写进任务描述。这是最省钱的一条——含糊描述导致的返工,是最贵的浪费。
- 给任务设合理的时限。简单任务别用默认的 7200 秒,600~1800 秒往往够用,能早点掐掉跑飞的轮次。
- 短活优先用 Agent 引擎。信息整合、接口调用、快速查询,用 Agent 比用循环执行省得多。
- 权重别乱给高分。只有真正重要的 1~2 个任务配高权重,其余保持低权重,避免"精力均摊"变成"精力浪费"。
- 把长任务拆小。一个"边做边验收"的拆解,比一个漫长的巨任务更省钱:早了结、早止损。
- 定期看"按角色花费分布"。找出最费钱的角色,优化它的提示词或改用更省的模型。
- 把重复性的活固化成模板。提示词模板固定后,AI 不用每次"重新理解需求",token 消耗会明显下降。
- 善用缓存。缓存读的单价只有普通输入的 1/50。稳定的上下文更容易命中缓存。
- 不要把项目晾在"运行中"却没事干。任务做完就让它进入空闲等待,而不是让它在 task 轮里反复空转。
- 及时处理人工节点。节点长时间挂起会拖慢进度、拉长项目周期,间接推高总成本。
- 预算预警一响就评估。到 80% 时看一眼"按天分布",判断是该补钱还是该收一收。
- 给预算科目分好类。把 token、第三方接口、算力分开记账,才知道钱到底花在哪一类上。
- 降低失败率。每一次连续失败都会走到"降级→升级",多花好几轮钱。稳定的外部接口和凭据能省不少。
- 不要给不重要的任务配高优先级。P0 会挤占其他人的排班,把紧急留给真紧急。
- 阶段性归档已完成目标。目标树保持干净,AI 的每次 review 都会更快、更省钱。
附录 E · 设计依据摘录
本手册的机制描述,来自以下几份正式文档;写"为什么这么设计"时可直接引用。它们也是产品后续演进的方向依据。
| 主题 | 依据文档 | 关键点 |
|---|---|---|
| 调度与轮次 | auto-ops 调度与轮次(分卷 04) | 时间片 + 轮次制;默认 10 个时间片;review 默认 20 轮;单轮默认 7200 秒;接力与完成标记 |
| 日志 / 人工 / 预算 / 时限 | auto-ops 日志人工预算时限(分卷 05) | L0–L3 自主级别;红黄绿三通道;双签复核;SLA 升级链;预算 80% 预警、超限熔断;豁免期默认 2 天 |
| 分析 / 对话 / 目标 / 计费 | auto-ops 分析对话目标治理与计费(分卷 06) | token 单价(输入 1 元/M、输出 2 元/M、缓存读 0.02 元/M);目标树 KR 加权达成率;权衡权重归一化 |
| 接口契约 | autoops 调度与轮次 API 文档、autoops 人工预算与审计 API 文档 | 生命周期、任务、轮次、human-tasks、budget/state、billing 等端点的字段与语义 |
本手册用三种标签标注能力现状:已上线 表示前后端都能用;部分可用 表示后端有、界面入口弱或需特定条件;规划中 表示设计在案、尚未开发。你在实际界面看到的功能,以界面为准。